随着大家对大数据分析越来越感兴趣,软件供应商Revolution Analytics改进了其R语言统计功能旗舰产品,使它能够与Hadoop数据处理平台运行。
这个新的Revolution R Enterprise 7(RRE 7)还能够使R在Teradata数据库内运行。
R语言提供了一种方法来对一组数据运行常用统计测试(例如线性和非线性建模、时间序列分析、分类和聚类),通常结果是以图形的形式出现。
R越来越多地用于复杂的数据分析,即那些超出标准商业智能程序包范围的数据分析。Revolution Analytics公司预计全世界有超过200万人在使用R。
RRE7包含R算法库——可以跨多个节点并行运行,这与Hadoop管理大数据集的方式相同。RRE7可以被添加到Cloudera CDH3和CDH4 Hadoop发行版,以及Hortonworks数据平台1.3。
这个新的R库保护最常用的统计和预测分析算法,用于数据处理、数据采样、描述性统计、统计测试、数据可视化、仿真、机器学习和预测模型等任务。
通过分析节点内的数据,而不是移动数据到其他位置进行分析,基于R的数据分析可以更快地进行。它还允许对一整组数据进行分析,而不是数据的子集或者摘要--企业数据仓库(EDW)通常是采用这样的方式。
Revolution Analytics希望将R加入到Hadoop和Teradata数据库可以拓宽该语言的使用范围。该公司还设计了一个新的工作流程界面,其中不需要知道如何部署特定的R算法。这缓解了使用Java或者其他语言编程R的麻烦,让其在Hadoop平台运行。
除了支持这些新的平台,RRE7还采用了一些新的算法和流程。其一是建立Decision Forests的模型集,Decision Forests是用于预测未来结果的机器学习技术。新的Stepwise Regression功能还可以帮助我们自动化选择用于预测模型中最重要的变量。新的Decision Tree可视化可以提供图形化的方式来描述数据集内复杂的关系和相关性。
华为行业数字化转型方法论白皮书2019下载,数字化转型是指产业与数字技术全面融合,提升效率的经济转型过程。
《中国数字经济发展与就业白皮书(2019年)》下载(信通院),2003-2018 年,我国数字经济增速显著高于同期GDP增速,产业数字化部分对数字经济增长的贡献度高达86.4%。
上交所上市公司海量数据昨晚发布了2019年半年度报告。报告显示,海量数据上半年实现营收2.28亿元,同比下降12.41%。
今天的大数据分析市场与几年前的市场截然不同,正是由于海量数据的暴增,未来十年,全球各行各业都将发生变革、创新和颠覆。
如何才能确保人们的医疗保健需求得到满足,不断提升生活质量?
【聚焦搜索,数智采购】2021第一届百度爱采购数智大会即将于5月28日在上海盛大开启!
本次大会上,紫晶存储董事、总经理钟国裕作为公司代表,与中国—东盟信息港签署合作协议
XEUS统一存储已成功承载宣武医院PACS系统近5年的历史数据迁移,为支持各业务科室蓬勃扩张的数据增量和访问、调用乃至分析需求奠定了坚实基础。
大兆科技全方面展示大兆科技在医疗信息化建设中数据存储系统方面取得的成就。
双方相信,通过本次合作,能够使双方进一步提升技术实力、提升产品品质及服务质量,为客户创造更大价值。